메뉴

#AI 학습

HN
Hacker News 2일 전
IMP 7

AI 학습용 희귀 도서, 산산조각 나다

AI 개발사들이 모델 학습 데이터를 확보하기 위해 역사적 가치가 있는 희귀 도서와 고서를 물리적으로 파괴(해체)하고 있습니다. 디지털화 과정에서 페이지를 뜯어내는 방식이 사용되는데, 이는 인류의 소중한 지식 유산을 훼손한다는 윤리적 비판을 받고 있습니다. 고도화된 AI 모델 개발을 위해 고품질 텍스트 데이터에 대한 기업들의 탐욕적인 수요가 빚어낸 부작용으로 해석됩니다.

데이터 수집 윤리 AI 학습
HN
Hacker News 15일 전
IMP 8

삼성, AI 학습 거부 시 헬스 데이터 영구 삭제 예고

삼성전자가 새로운 AI 모델 학습에 개인 건강 데이터를 활용하도록 강제하고 있으며, 동의하지 않을 경우 데이터를 영구 삭제하겠다고 경고하고 있습니다. 사용자 데이터가 내부 직원 및 외부 인력에 의해 검토될 수 있다는 점 때문에 강력한 데이터 활용 동의와 개인정보 보호 논란이 예상됩니다. 이는 AI 기반 헬스케어 서비스 고도화를 위한 기업의 데이터 확보 경쟁이 극단적인 형태로 나타난 중요한 사례입니다.

개인정보보호 데이터 활용 삼성전자
TC
TechCrunch AI 27일 전
IMP 8

클라우드플레어, AI 기업의 콘텐츠 무단 수집 제한 예정

클라우드플레어가 2026년 9월부터 검색과 AI 학습을 동시에 수행하는 크롤러의 접근을 기본적으로 차단하여 퍼블리셔의 지식재산권을 보호합니다. 또한 AI가 콘텐츠를 활용해 가치를 창출할 때 퍼블리셔가 수익을 분배받을 수 있는 '페이 퍼 유즈(Pay Per Use)' 모델을 도입했습니다. 이는 웹 생태계의 지속 가능성을 보장하고 AI 기업들에게 콘텐츠 사용에 대한 정당한 대가를 지불하도록 유도하는 중요한 변화입니다.

클라우드플레어 AI 학습 저작권
SG
r/singularity 78일 전
IMP 8

저커버그, AI 학습 위해 대규모 저작권 침해 지휘

메타(Meta)와 마크 저커버그(Mark Zuckerberg) CEO가 소설가 스콧 투로우(Scott Turow) 및 5개 출판사로부터 제소당했습니다. 원고 측은 메타가 AI 시스템 학습을 위해 수백만 권의 저작물을 불법으로 복제했다고 주장합니다. 특히 저커버그가 이러한 대규모 저작권 침해를 직접 승인하고 장려했다는 점이 이번 소송의 핵심입니다.

저작권 메타 AI 학습
TD
The Decoder 88일 전
IMP 6

챗GPT의 고블린 폭주, AI 학습의 근본적 문제 지적

OpenAI의 GPT-5.1 이후 모델부터 응답에 고블린 등 가상의 생물이 언급되는 기현상이 발생했습니다. 원인은 '너디(Nerdy)' 성격 모드 학습 과정에서 보상 신호가 생물 비유를 선호하는 피드백 루프를 만들었기 때문입니다. 이 사례는 미세한 학습 보상이 AI 모델의 전반적인 동작에 예기치 않은 큰 영향을 미칠 수 있음을 보여줍니다.

OpenAI AI 학습 보상 모델